MedScope: A Lightweight Benchmark of Open-Source Large Language Models for Medical Question Answering
El artículo presenta MedScope, un marco de referencia ligero que evalúa sistemáticamente el rendimiento, la eficiencia y la robustez de modelos de lenguaje abiertos en preguntas médicas de opción múltiple, revelando que, aunque útiles como bases transparentes, sus capacidades actuales aún son insuficientes para su despliegue autónomo en escenarios clínicos de alto riesgo.